IT之家 08-27 07:01

阿里通义 Qwen3.8-Flash(Next)发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9

📌 一句话:阿里开源千亿参数MoE大模型,训练成本骤降至前代九分之一

💡 3个要点

  • 1250亿参数混合专家架构:采用MoE设计,每次推理仅激活部分专家,大幅降低计算开销

  • 训练成本骤降90%:对比前代同规模模型,训练资源消耗仅为九分之一,性价比极高

  • 全面开源可商用:采用Apache 2.0协议,企业和个人可免费使用,降低AI应用门槛

📖 背景

MoE(Mixture of Experts)混合专家架构通过动态激活不同"专家"网络,能在保持大参数量的同时显著降低计算成本。阿里自Qwen系列开源以来,持续推进大模型平民化战略,此次成本控制突破意味着更多开发者能在有限资源下训练和部署顶级AI能力。

💭 点评

训练成本降低90%不只是技术优化,更是AI民主化的里程碑。当千亿参数模型的训练从"大厂专属"变成"人人可为",整个行业的游戏规则都在被改写。阿里押注开源生态的战略眼光狠辣——用低成本换大市场,用开源换生态主导权。这一仗,中国AI厂商没有缺席。

码头码农 - 微信搜索关注